Benchmarking Speech Recognition Models for Medical Consultations in Latin American Spanish: A Comparative Evaluation with Fine-Tuning
यह अध्ययन लैटिन अमेरिकी स्पेनिश चिकित्सा परामर्शों पर दस स्पीच-टू-टेक्स्ट मॉडलों का बेंचमार्किंग करता है, जिसमें यह पाया गया कि हालांकि व्हिस्पर लार्ज v3 (Whisper Large v3) को फाइन-ट्यून करने से यह अपने वैनिला संस्करण से आगे नहीं निकल पाया, फिर भी इसने प्रमुख मेट्रिक्स पर अन्य ओपन-सोर्स और क्लोज्ड-सोर्स मॉडलों को पछाड़ दिया, जिससे इसे इस संदर्भ में एआई मेडिकल स्क्राइब्स के लिए इष्टतम ओपन-सोर्स समाधान के रूप में स्थापित किया गया है।